梁神变牢梁的原因找到了!疑似 DeepSeek 发错模型,HF配置和API后台紧急切换
梁神变牢梁的原因找到了!疑似 DeepSeek 发错模型,HF配置和API后台紧急切换DeepSeek-v4-pro-0813 正式上线,两极分化的口碑却让人摸不着头脑。一边,是疯狂刷屏的评测夯爆了:多项 Agent 测试逼近 Fable 5,被认为是又一次前沿模型的“核弹级”更新;另一边,却是不少深夜忠实开发者直摇头:吐槽涨价、模型能力不及预期,实测体感甚至不如之前的小模型……
搜索
DeepSeek-v4-pro-0813 正式上线,两极分化的口碑却让人摸不着头脑。一边,是疯狂刷屏的评测夯爆了:多项 Agent 测试逼近 Fable 5,被认为是又一次前沿模型的“核弹级”更新;另一边,却是不少深夜忠实开发者直摇头:吐槽涨价、模型能力不及预期,实测体感甚至不如之前的小模型……
背后由清华大学、北京大学等一众机构支持的 Agent Memory Leaderboard(中文名「记忆之巅排行榜」)放出了首期成绩,目前该项目上榜 Huggingface Spaces Trending 首屏。
成立不到三年,首颗AI芯片进入量产,又拿下1.3亿美元B轮融资,Acrab正在成为亚洲AI芯片市场里最值得关注的新贵之一。据DealStreetAsia报道,这家总部位于新加坡的AI计算基础设施公司近日完成B轮融资,Vertex Growth等机构参与投资。
过去一年,编程 Agent 的能力大幅提升,软件工程师对它们的要求也比以往任何时候都高,但上下文窗口的大小却基本停滞不前——一年前,一百万个 token 大致就是最先进的水平,如今依然如此。随着我们逐渐进入 Agent 日常处理 Monorepo(单体仓库)级任务的世界,将越来越多的信息塞进模型那固定的上下文限制中,这种需求已经变成了一项实实在在的全职工程任务。
视频模型这个月很热闹。7 月 31 日,MiniMax H3 和字节跳动 Seedance 2.5 同日发布。3 天后,MiniMax H3 正式开源;8 月 7 日,Seedance 2.5 开放 api。模型越来越好了,但产品能把它用好吗?
距离 3.6 Flash 发布才过去 3 周,Google 又端上了 Gemini 3.7 Flash。刚刚接掌 Google DeepMind 的 Koray Kavukcuoglu 发文介绍,这是新一代面向 Coding 和 Agent 工作流的主力模型,首发价格只有 Gemini 3.6 Flash 原始价格的一半。
MiniMax 过去一年的 agent 实践,从一个内部飞书 bot 开始,演化成了桌面应用 MiniMax Code,最终形成了一个训练-服务的闭环:模型在自己的 harness 里训练,通过 harness 服务用户,用户行为变成训练信号反哺下一个模型。这个闭环是模型公司设计 Agent 的核心逻辑。
对 Agent 来说,这种长期记忆能力,正逐渐成为影响实际可用性的一项基础能力。今天,Agent Memory Leaderboard(AML,记忆之巅排行榜)正式发布首期结果。
当基础模型随时可能吃掉应用层,创业公司还剩下多少空间?热钱涌入 Agent 和具身智能,高估值究竟由什么支撑?如果技术兑现的速度赶不上资本预期,又会由谁承担代价?围绕这些问题,Alphaist 创始人陈哲与蓝驰创投管理合伙人陈维广在 AGI Playground 2026 上展开了一场对谈。
MiraDay 正是为了解决这个问题而诞生的,作为科锐国际孵化的一款 Talent Intelligence 产品,MiraDay 面向企业内部招聘团队和猎头公司,重点服务高管和关键技术人才招聘。它希望让 AI 承担数据搜集、信息整理和重复工作,让人类把更多精力放在人才判断、沟通和关系建立上。